사진·스크린샷·스캔 PDF에서 이미지 텍스트 추출과 PDF OCR을 사용자 기기에서 처리합니다. 선택 가능한 텍스트가 있는 PDF 페이지는 OCR 대신 텍스트 레이어를 직접 읽습니다.
JPG, PNG, WebP, BMP, PDF · 원본 파일은 MISCLAND 서버로 업로드되지 않습니다.
아닙니다. 선택한 이미지와 PDF 원본은 서버로 업로드하지 않고 현재 브라우저 메모리에서 처리합니다.
OCR 계산도 PaddleOCR.js와 WebAssembly를 이용해 사용자의 PC·모바일 기기에서 실행합니다. MISCLAND 서버는 정적 OCR 엔진과 모델 파일을 전달할 뿐, 문서 내용이나 OCR 결과를 받거나 저장하지 않습니다.
PDF 페이지에 선택 가능한 텍스트가 이미 있으면 PDF.js로 텍스트를 직접 추출합니다. 이 방식은 OCR보다 빠르고 원문 정확도도 높습니다.
텍스트 레이어가 없는 스캔 페이지나 사진형 PDF만 브라우저에서 이미지로 렌더링한 뒤 OCR을 실행합니다. 한 PDF 안에 텍스트 페이지와 스캔 페이지가 섞여 있어도 페이지별로 자동 분기합니다.
한국어, 영어, 스페인어, 포르투갈어, 프랑스어, 독일어, 이탈리아어, 인도네시아어, 베트남어, 아랍어, 힌디어, 중국어 간체·번체, 일본어를 선택할 수 있습니다.
언어별로 적합한 PP-OCRv5 모바일 인식 모델을 사용합니다. 모델은 필요한 언어를 선택하고 실제 OCR을 시작할 때만 로드되며 브라우저 캐시를 활용합니다.
OCR은 원본 화질, 글자 크기, 기울기, 배경, 글꼴에 따라 오인식이 생길 수 있으므로 100% 정확도를 보장하지 않습니다.
선명한 인쇄 문서와 스캔본에서 가장 좋은 결과를 얻을 수 있습니다. 작은 글자가 많으면 고품질 모드를 사용하고, 흐린 흑백 문서는 문서 보정을 함께 사용해 보세요. 중요한 문서는 결과를 반드시 원본과 대조하세요.
네. WebAssembly와 Web Worker를 지원하는 최신 모바일 브라우저에서 사용할 수 있습니다.
OCR은 사용자 기기의 메모리와 연산 자원을 사용하므로 저사양 기기나 매우 큰 문서에서는 시간이 오래 걸릴 수 있습니다. 모바일에서는 파일 수·총 용량·PDF 페이지 수·이미지 해상도에 더 낮은 안전 한도를 자동 적용합니다.